即時快訊
【專家觀點】AI 沒有殺死軟體業,而是正在重寫軟體:Agent 時代的 IT 產業大洗牌 佛州棕櫚灣市自主開發AI 應對數據風險與採購挑戰 科技巨頭紛祭API存取限制 AI代理戰爭掀新篇章 2027韓國消費趨勢出爐:「領航者」與「倦怠社會」成關鍵 聯準會新主席凱文·沃什首度升息 強硬獨立態度獲市場認可 美國股市第四季面臨多重逆風 聯準會緊縮與地緣政治添變數 美半導體龍頭應用材料攜手 Besi 強化先進封裝共建 AI 晶片生態 美國信貸市場浮現四大趨勢 銀行應對挑戰需借鏡 日立製作所成日本首例 加入Linux基金會「Tokenomics」推動人工智慧價值評估 美國基金押注中國AI模型ETF 專家點名台積電等亞洲巨頭受惠
防範強大AI風險 Google DeepMind揭示控制路線圖
科技生活

·3 months ago·林昭衡
#Google DeepMind#AI安全#AI代理人#資安#控制路線圖
防範強大AI風險 Google DeepMind揭示控制路線圖
商傳媒|林昭衡/綜合外電報導
摘要

Google DeepMind 近日發布一份AI控制路線圖,旨在透過系統級安全措施及可信賴的AI監督者,監控並管理其強大AI代理人的行為,以防範潛在風險,強調AI安全正從哲學討論轉向資訊安全實踐。

Google DeepMind 近日發布一份 AI Control Roadmap(AI控制路線圖),旨在強化內部強大 AI 代理人的安全性與管理。這份藍圖強調,除了透過對齊(alignment,即訓練模型使其行為符合預期)來保障 AI 的方式外,還需增設系統級的安全機制,以全面防範潛在風險。

該控制路線圖的核心理念之一是透過可信賴的 AI 監督者,對 AI 代理人的推論過程、實際行動與執行計畫進行全面監控。這些控制措施將根據風險程度進行調整,對於低風險行為,可能僅需延遲審查;但對於具有潛在危險性的行動,則會實施即時阻擋。Google DeepMind 表示,此概念借鑒了資安領域的經驗,因為資安領域早已深知「即使是可信賴的系統,也可能遭受入侵」的教訓。

未來的 AI 代理人架構預計將結合多種安全元素,包括模型評估(model evals)、存取控制(access control)、稽核日誌(audit logs)、沙盒(sandboxing,即在隔離環境中執行)以及由 AI 監督其他 AI 的機制。為確保這些控制措施的有效性,Google DeepMind 也定義了具體的衡量指標:覆蓋率(監控的代理人流量比例)、召回率(捕獲不良行為的比例)以及反應時間(系統阻止不良行為的速度)。

此發展也反映了整個產業對 AI 安全的重視,例如 OpenAI 的 Dean Ball 已加入該公司,領導一個 Strategic Futures team(策略未來團隊),專注於前瞻 AI 政策的制定。這顯示 AI 安全的焦點正從抽象的哲學探討,轉向更具體的資訊安全實踐。


在 Google 搜尋的熱門報導中優先看到商傳媒
加入為 Google 偏好來源